Type: entity
Confidence: 0.80
Created: 2026-04-18
Updated: 2026-04-18
Tags: 技术AI推理引擎工具与框架

ONNX Runtime

概述

ONNX Runtime 是微软开源的跨平台机器学习推理加速器,支持 ONNX 格式模型的 GPU/CPU 自动选择执行,是 MinerUDocLayout-YOLO 等模型的推理引擎。

关键内容

核心特性

在 MinerU 中的使用

import onnxruntime as ort

session = ort.InferenceSession(
    "doclayout_yolo.onnx",
    providers=["CUDAExecutionProvider", "CPUExecutionProvider"]
)

input_tensor = img_normalized[np.newaxis, :]  # 添加 batch 维度
outputs = session.run(None, {"images": input_tensor})

通过 providers 列表指定优先级,优先使用 GPU 加速,不可用时自动降级到 CPU。

推理流程

  1. 加载 .onnx 模型文件创建 InferenceSession
  2. 预处理输入(归一化、添加 batch 维度)
  3. 调用 session.run() 执行推理
  4. 解析原始输出([1, num_predictions, 4+num_classes] 格式)
  5. 后处理(坐标还原、NMS、类别映射)

来源

相关